<!DOCTYPE html>
<html class="client-nojs vector-feature-language-in-header-enabled vector-feature-language-in-main-page-header-disabled vector-feature-page-tools-pinned-disabled vector-feature-toc-pinned-clientpref-0 vector-toc-not-available vector-feature-main-menu-pinned-disabled vector-feature-limited-width-clientpref-1 vector-feature-limited-width-content-enabled vector-feature-custom-font-size-clientpref-1 vector-feature-appearance-pinned-clientpref-0 skin-theme-clientpref-day vector-sticky-header-enabled" lang="de" dir="ltr"><head>
<meta charset="UTF-8">
<title>Validität</title>
<meta name="viewport" content="width=device-width, initial-scale=1.0">
<link rel="icon" type="image/png" href="./_res_/favicon.png">
<link rel="canonical" href="https://de.wikipedia.org/wiki/Validit%C3%A4t"> <link href="./_mw_/ext.cite.styles.css" rel="stylesheet" type="text/css">
<link href="./_mw_/ext.wikimediamessages.styles.css" rel="stylesheet" type="text/css">
<link href="./_mw_/skins.vector.icons.css" rel="stylesheet" type="text/css">
<link href="./_mw_/skins.vector.search.codex.styles.css" rel="stylesheet" type="text/css">
<link href="./_mw_/skins.vector.styles.css" rel="stylesheet" type="text/css">
<meta name="ResourceLoaderDynamicStyles" content="">
<link href="./_mw_/ext.gadget.citeRef.css" rel="stylesheet" type="text/css">
<link href="./_mw_/ext.gadget.defaultPlainlinks.css" rel="stylesheet" type="text/css">
<link href="./_mw_/ext.gadget.dewikiCommonHide.css" rel="stylesheet" type="text/css">
<link href="./_mw_/ext.gadget.dewikiCommonLayout.css" rel="stylesheet" type="text/css">
<link href="./_mw_/ext.gadget.dewikiCommonStyle.css" rel="stylesheet" type="text/css">
<link href="./_mw_/ext.gadget.dewikiDarkmode.css" rel="stylesheet" type="text/css">
<link href="./_mw_/ext.gadget.dewikiResponsive.css" rel="stylesheet" type="text/css">
<link href="./_mw_/ext.gadget.specialSearch.css" rel="stylesheet" type="text/css">
<link rel="stylesheet" type="text/css" href="./_mw_/site.styles.css">
<link rel="stylesheet" type="text/css" href="./_mw_/noscript.css">
<link rel="stylesheet" type="text/css" href="./_res_/footer.css">
<link rel="stylesheet" type="text/css" href="./_res_/vector-2022.css">
</head>
<body class="skin--responsive skin-vector skin-vector-search-vue mediawiki ltr sitedir-ltr mw-hide-empty-elt ns-0 ns-subject page-Validität rootpage-Validität skin-vector-2022 action-view">
<div class="mw-page-container">
<div class="mw-page-container-inner">
<div class="mw-content-container">
<main id="content" class="mw-body">
<header class="mw-body-header vector-page-titlebar">
<h1 id="firstHeading" class="firstHeading mw-first-heading"><span class="mw-page-title-main">Validität</span></h1>
</header>
<a id="top"></a>
<div id="bodyContent" class="vector-body ve-init-mw-desktopArticleTarget-targetContainer" aria-labelledby="firstHeading" data-mw-ve-target-container="">
<div id="contentSub">
<div id="mw-content-subtitle"></div>
</div>
<div id="mw-content-text" class="mw-body-content mw-content-ltr" lang="de" dir="ltr"><div class="mw-content-ltr mw-parser-output" lang="de" dir="ltr"><p><b>Validität</b> (<span style="font-style:normal;font-weight:normal"><a href="Latein" title="Latein">lateinisch</a></span> <span lang="la-Latn" style="font-style:italic"><i>validus</i></span> „kräftig“ „wirksam“; <span style="font-style:normal;font-weight:normal"><a href="Englische_Sprache" title="Englische Sprache">englisch</a></span> <span lang="en-Latn" style="font-style:italic"><i>validity</i></span>; auch: <b>Gültigkeit</b>) ist (neben der <a href="Reliabilit%C3%A4t" title="Reliabilität">Reliabilität</a> und der <a href="Objektivit%C3%A4t_(Testtheorie)" title="Objektivität (Testtheorie)">Objektivität</a>) ein Gütekriterium für <a href="Modell" title="Modell">Modelle</a>, <a href="Messung" title="Messung">Mess-</a> oder <a href="Test" title="Test">Testverfahren</a>.
</p><p>Validität bezeichnet in der <a href="Empirie" title="Empirie">Empirie</a> die inhaltliche Übereinstimmung einer empirischen Messung mit einem logischen Messkonzept. Allgemein ist dies der Grad an Genauigkeit, mit der dasjenige Merkmal tatsächlich gemessen wird, das gemessen werden soll.<sup id="cite_ref-1" class="reference"><a href="#cite_note-1"><span class="cite-bracket">[</span>1<span class="cite-bracket">]</span></a></sup>
Bezüglich Modellen und <a href="Hypothese" title="Hypothese">Hypothesen</a> bezeichnet Validität die Übereinstimmung von <a href="Prognose" title="Prognose">Prognose</a> respektive <a href="Schlussfolgerung" title="Schlussfolgerung">Schlussfolgerungen</a> und Daten.
</p><p>Dabei unterscheidet man zwischen einem <i>Repräsentationsschluss</i> (wenn das Testverhalten repräsentativ für Gesamtverhalten ist) und einem <i>Korrelationsschluss</i> (wenn das Verhalten im Test mit dem Verhalten außerhalb der Testsituation korreliert).<sup id="cite_ref-2" class="reference"><a href="#cite_note-2"><span class="cite-bracket">[</span>2<span class="cite-bracket">]</span></a></sup> Je nachdem, welche Variable als Kriterium für das Verhalten außerhalb der Testsituation verwendet wird, unterscheidet man zwischen <i>inhaltlicher, prädiktiver</i> oder <i>Konstruktvalidität</i>.<sup id="cite_ref-3" class="reference"><a href="#cite_note-3"><span class="cite-bracket">[</span>3<span class="cite-bracket">]</span></a></sup>
</p>
<div class="mw-heading mw-heading2"><h2 id="Validität_als_Gütekriterium_für_Messinstrumente"><span id="Validit.C3.A4t_als_G.C3.BCtekriterium_f.C3.BCr_Messinstrumente"></span>Validität als Gütekriterium für Messinstrumente</h2></div>
<p>Die Validität gehört zu den sogenannten <a href="G%C3%BCtekriterien_psychodiagnostischer_Verfahren" class="mw-redirect" title="Gütekriterien psychodiagnostischer Verfahren">Hauptgütekriterien</a> für <a href="Messger%C3%A4t" title="Messgerät">Messinstrumente</a>. Sie ist ein Maß dafür, ob die bei der Messung erzeugten Daten wie beabsichtigt die zu messende Größe repräsentieren. Nur dann können die Daten sinnvoll interpretiert werden.
</p><p>Neben der Validität gehören die <a href="Objektivit%C3%A4t_(Testtheorie)" title="Objektivität (Testtheorie)">Objektivität</a> (Unabhängigkeit der Ergebnisse von den Messbedingungen) und die <a href="Reliabilit%C3%A4t" title="Reliabilität">Reliabilität</a> (Zuverlässigkeit, formale Genauigkeit der Messung) zu den drei Haupt-Gütekriterien. Sie bauen aufeinander auf: Ohne Objektivität keine Reliabilität, ohne Reliabilität keine Validität.
</p>
<dl><dd><i>Beispiel: Wenn ein Test die Fahrtauglichkeit vorhersagen soll, werden entsprechende Aufgaben (z. B. zur Konzentration, Wahrnehmung, Sensumotorik, Intelligenz) zusammengestellt, die nach der Durchführung einen Testwert liefern. Dieser muss objektiv und zuverlässig sein. Validität betrifft die Frage, ob er tatsächlich die Fahrtauglichkeit vorhersagt und z. B. Personen mit entsprechendem Risiko identifiziert. Trotz vorliegender Objektivität und Zuverlässigkeit muss die Validität nicht gegeben sein, z. B. wenn gemessene Merkmale nicht repräsentativ für die Fahrtauglichkeit sind.</i></dd></dl>
<p>Es gibt verschiedene Aspekte der Validität und zugeordnete Mess- und Schätzverfahren.
</p>
<div class="mw-heading mw-heading3"><h3 id="Validität_als_Gütekriterium_für_psychologische_Tests"><span id="Validit.C3.A4t_als_G.C3.BCtekriterium_f.C3.BCr_psychologische_Tests"></span>Validität als Gütekriterium für psychologische Tests</h3></div>
<p>Vor allem für <a href="Psychologischer_Test" title="Psychologischer Test">psychologische Tests</a> finden diese Gütekriterien als Bewertungskriterien der Qualität Anwendung. Ein Test muss so konstruiert sein, dass Durchführung, Auswertung und Interpretation unabhängig vom Testleiter oder den Untersuchungsbedingungen sind (Objektivität) sowie das Testergebnis sich auch mit dem gleichen oder einem vergleichbaren Test bestätigt (Reliabilität). Die Validität oder Gültigkeit ist darauf bezogen, dass z. B. durch einen Intelligenztest wirklich Aspekte der <a href="Intelligenz" title="Intelligenz">Intelligenz</a> gemessen werden und diese Messung eine Vorhersage der Leistungsfähigkeit im realen Leben (z. B. Ausbildungserfolg oder Berufserfolg) erlaubt. Solche Vorhersagen sind messungsbedingt mit einem Fehler versehen und nur Wahrscheinlichkeitsaussagen – zugleich wird an einigen Inhalten auch Kritik geübt, vgl. z. B. <a href="Kritik_am_Intelligenzbegriff" title="Kritik am Intelligenzbegriff">Kritik am Intelligenzbegriff</a>.
</p>
<div class="mw-heading mw-heading2"><h2 id="Formen_und_Aspekte_der_Validität"><span id="Formen_und_Aspekte_der_Validit.C3.A4t"></span>Formen und Aspekte der Validität</h2></div>
<p>In ihren <i>Technical recommendations for psychological tests and diagnostic techniques</i> (1954) schlug die <a href="American_Psychological_Association" title="American Psychological Association">American Psychological Association</a> vier Arten der Validität vor, diese sind <i>Inhaltsvalidität</i>, <i>Konstruktvalidität</i> und <i>prognostische</i> sowie <i>diagnostische Kriteriumsvalidität</i>, von denen „historisch und praktisch gesehen […] die kriteriumsbezogene Validität der bedeutsamste Aspekt“<sup id="cite_ref-4" class="reference"><a href="#cite_note-4"><span class="cite-bracket">[</span>4<span class="cite-bracket">]</span></a></sup> ist. „Die Übereinkunft durch ein Rating ist wie alle Übereinkünfte nicht etwas Abgeschlossenes, sondern kann einem ständigen Wandel unterworfen sein. […] Es bleibt dabei jedem Testinterpreten überlassen, dieses Kriterium anzuerkennen oder zu verwerfen bzw. nach einem besseren zu suchen.“<sup id="cite_ref-5" class="reference"><a href="#cite_note-5"><span class="cite-bracket">[</span>5<span class="cite-bracket">]</span></a></sup>
</p>
<div class="mw-heading mw-heading3"><h3 id="Inhaltsvalidität"><span id="Inhaltsvalidit.C3.A4t"></span>Inhaltsvalidität</h3></div>
<div class="hauptartikel" role="navigation"><span class="hauptartikel-pfeil" title="siehe" aria-hidden="true" role="presentation">→ </span><i><span class="hauptartikel-text">Hauptartikel</span>: <a href="Inhaltsvalidit%C3%A4t" title="Inhaltsvalidität">Inhaltsvalidität</a></i></div>
<p>Inhaltsvalidität (engl. <i><span lang="en">content validity</span></i>) wird angenommen, wenn ein Verfahren zur Messung eines bestimmten <a href="Konstrukt" title="Konstrukt">Konstrukts</a> oder <a href="Pers%C3%B6nlichkeitseigenschaft" title="Persönlichkeitseigenschaft">Merkmals</a> die bestmögliche <a href="Operationalisierung" title="Operationalisierung">Operationalisierung</a> dieses Konstrukts ist. Das ist zum Beispiel bei Interessen- und Kenntnistests der Fall: Eine Klassenarbeit oder Führerscheinprüfung repräsentieren direkt die zu messenden Fähigkeiten. Daher spricht man auch von <i>logischer</i> oder <i>trivialer Validität</i>. Ob Inhaltsvalidität gegeben ist oder nicht, entscheiden Experten per Rating.
</p>
<div class="mw-heading mw-heading3"><h3 id="Konstruktvalidität"><span id="Konstruktvalidit.C3.A4t"></span>Konstruktvalidität</h3></div>
<div class="hauptartikel" role="navigation"><span class="hauptartikel-pfeil" title="siehe" aria-hidden="true" role="presentation">→ </span><i><span class="hauptartikel-text">Hauptartikel</span>: <a href="Konstruktvalidit%C3%A4t" title="Konstruktvalidität">Konstruktvalidität</a></i></div>
<p>Unter dem Begriff <a href="Konstrukt" title="Konstrukt">Konstrukt</a> werden theoretische Eigenschaftsdimensionen (<a href="Latente_Variablen" class="mw-redirect" title="Latente Variablen">latente Variablen</a>) verstanden. Konstruktvalidität bezieht sich auf die Zulässigkeit von Aussagen aufgrund der Operationalisierung über das gesamte dahinter liegende Konstrukt. Dies ist in der Regel dann der Fall, wenn der Bedeutungsumfang des Konstruktes vollständig, präzise und nachvollziehbar abgebildet ist. Als empirische Indikatoren der Konstruktvalidität gelten die <i>konvergente</i> sowie <i>diskriminante</i> (oder auch: <i>divergente</i>) <i>Validität</i>:
</p>
<dl><dt><a href="Konvergenzvalidit%C3%A4t" title="Konvergenzvalidität">Konvergenzvalidität</a></dt>
<dd>Die Messdaten von Testverfahren, die dasselbe Konstrukt abbilden, müssten hoch miteinander <a href="Korrelation" title="Korrelation">korrelieren</a>.</dd>
<dt><a href="Diskriminanzvalidit%C3%A4t" title="Diskriminanzvalidität">Diskriminanzvalidität</a></dt>
<dd>Die Messdaten von Testverfahren, die verschiedene Konstrukte abbilden, sollten nur gering miteinander korrelieren (sofern die Konstrukte auch tatsächlich voneinander unabhängig sind).</dd></dl>
<p>Sowohl konvergente als auch diskriminante Validität müssen gegeben sein, um einen vollständigen Nachweis der Konstruktvalidität zu gewährleisten. Das empirische Vorgehen bei der konvergenten und diskriminanten Validität sind Spezialfälle der Kriteriumsvalidität.
</p><p>Bei der <a href="Multitrait-Multimethod-Matrix" title="Multitrait-Multimethod-Matrix"><i>Multitrait-Multimethod-Analyse</i></a> werden die konvergente Validität und die diskriminante Validität anhand einer einzigen Stichprobe miteinander verglichen. Dabei wird verkürzt gesagt erwartet, dass die konvergente Validität größer ist als die diskriminante Validität.
</p><p><b>Faktoren für eine verminderte Konstruktvalidität</b> können sein:<sup id="cite_ref-Krauth_2000_6-0" class="reference"><a href="#cite_note-Krauth_2000-6"><span class="cite-bracket">[</span>6<span class="cite-bracket">]</span></a></sup>
</p>
<ul><li>vage Definition des Konstruktes</li>
<li><i><span lang="en">mono-operation bias</span></i>: nur ein Aspekt des Konstruktes wird untersucht</li>
<li><i><span lang="en">mono-method bias</span></i>: nur eine Methode wird zur Operationalisierung des Konstruktes verwendet</li>
<li>Hypothesenraten (<a href="Hawthorne-Effekt" title="Hawthorne-Effekt">Hawthorne-Effekt</a>)</li>
<li><a href="Soziale_Erw%C3%BCnschtheit" title="Soziale Erwünschtheit">soziale Erwünschtheit</a></li>
<li>Erwartungen des Versuchsleiters (<a href="Rosenthal-Effekt" title="Rosenthal-Effekt">Rosenthal-Effekt</a>)</li>
<li>Auslassen relevanter Faktorstufen</li>
<li>mehr als eine <a href="Unabh%C3%A4ngige_Variable" class="mw-redirect" title="Unabhängige Variable">unabhängige Variable</a> ist wirksam (siehe <a href="Konfundierungseffekt" class="mw-redirect" title="Konfundierungseffekt">Konfundierungseffekt</a>)</li>
<li>Wechselwirkung zwischen Messung und Behandlung</li>
<li>eingeschränkte Generalisierbarkeit auf ähnliche Variablen</li></ul>
<div class="mw-heading mw-heading3"><h3 id="Kriteriumsvalidität"><span id="Kriteriumsvalidit.C3.A4t"></span>Kriteriumsvalidität</h3></div>
<p>Kriteriumsvalidität bezieht sich auf den Zusammenhang zwischen den Ergebnissen des Messinstruments und einem empirischen Kriterium (Schnell, Hill & Esser, 2005, S. 155). Zum Beispiel: Ein Forscher untersucht den Zusammenhang seines neuen Intelligenztests mit den Schulnoten der Probanden, um die Gültigkeit seines Tests zu prüfen. Von „innerer (Kriteriums)validität“ wird dabei dann gesprochen, wenn als Kriterium ein anderer, als valide anerkannter Test herangezogen wird. Sofern als Kriterium ein objektives Maß (zum Beispiel psychophysiologische Maße oder ökonomische Größen) oder ein Expertenrating herangezogen wird, wird von <i>äußerer (Kriteriums)validität</i> gesprochen. Auch lässt sich unterscheiden nach dem Zeitpunkt, zu dem Übereinstimmung mit dem Kriterium vorliegen soll:
</p>
<dl><dt>Diagnostische Validität / Übereinstimmungsvalidität (<i><span lang="en">concurrent validity</span></i>)</dt>
<dd>Das Außenkriterium, das bereits valide sein muss (z. B. ein anderer Test), wird zeitgleich mit dem zu validierenden Messinstrument den gleichen Versuchspersonen dargeboten. Die Ergebnisse der beiden Messinstrumente werden <a href="Korrelation" title="Korrelation">korreliert</a>. Die Höhe der Korrelation ist das Maß für die Übereinstimmungsvalidität. Das Vorgehen zur Ermittlung der konvergenten und der diskriminanten Testvalidität sind Spezialfälle dieser Kategorie.</dd></dl>
<dl><dt>Prognostische Validität / Vorhersagevalidität (<span lang="en"><i>predictive validity</i></span>)</dt>
<dd>Die Messdaten werden zu einem Zeitpunkt erhoben, der vor der Erhebung des Außenkriteriums liegt. Im Unterschied zur Übereinstimmungsvalidität liegt bei der Bestimmung der Vorhersagevalidität das <a href="Prognoseintervall" title="Prognoseintervall">Prognoseintervall</a> zwischen den beiden Messungen. So kann der Grad bestimmt werden, in dem die Messdaten das Kriterium vorhersagen. Zum Beispiel kann im Rahmen eines <a href="Assessment-Center" title="Assessment-Center">Assessment-Centers</a> eine Prognose für beruflichen Erfolg gestellt werden, oder aus der Leistung in einem <a href="Intelligenztest" title="Intelligenztest">Intelligenztest</a> wird der spätere Schulerfolg vorhergesagt. Ein Test erfüllt die Vorhersagevalidität, wenn seine Vorhersagen hoch mit dem tatsächlich später eingetretenen Ergebnis korrelieren.</dd></dl>
<div class="mw-heading mw-heading3"><h3 id="Augenscheinvalidität"><span id="Augenscheinvalidit.C3.A4t"></span>Augenscheinvalidität</h3></div>
<p>Augenscheinvalidität, auch als <i><span lang="en">face validity</span></i> bezeichnet, hängt davon ab, ob ein Messinstrument auch Laien plausibel erscheint. Augenscheinvalidität sagt nichts über die tatsächliche Validität, also die Inhalts-, Kriteriums- und Konstruktvalidität aus, sondern bestimmt über die Akzeptanz für ein Messverfahren. Auch sehr wenig valide Messinstrumente (wie z. B. unstrukturierte Einstellungsinterviews) erfreuen sich hoher Augenscheinvalidität und werden in der Praxis deshalb häufig eingesetzt.
</p>
<div class="mw-heading mw-heading2"><h2 id="Validität_von_Aussagen_über_Kausalzusammenhänge"><span id="Validit.C3.A4t_von_Aussagen_.C3.BCber_Kausalzusammenh.C3.A4nge"></span>Validität von Aussagen über Kausalzusammenhänge</h2></div>
<p>Aufbauend auf den auf einzelne Konstrukte bezogenen Operationalisierungen ziehen in den meisten <a href="Empirie" title="Empirie">empirischen</a> Studien Forscher erst in der statistischen Auswertung und danach im Hinblick auf ihre <a href="Kausalit%C3%A4t" title="Kausalität">Kausalhypothesen</a> Schlussfolgerungen über Ursache-Wirkungs-Zusammenhänge. Die Begriffe der <i>statistischen</i>, <i>internen</i> und <i>externen Validität</i> beziehen sich auf das Zustandekommen, die Gültigkeit und die Übertragbarkeit dieser (<a href="Induktion_(Philosophie)" title="Induktion (Philosophie)">induktiven</a>) Schlüsse. Der Validitätsgrad dieser Schlüsse lässt sich jeweils nur diskutieren und abschätzen, niemals beweisen, und es ist darum – wie gehabt – sinnvoller, eher vom Validitätsgrad zu sprechen als vom Vorhandensein (oder Nicht-Vorhandensein) dieser Validitätsformen.
</p>
<div class="mw-heading mw-heading3"><h3 id="Statistische_Validität"><span id="Statistische_Validit.C3.A4t"></span>Statistische Validität</h3></div>
<p>Für Aussagen oder in empirischen Studien gezogene Schlussfolgerungen (in der Regel über Ursache-Wirkungs-Verhältnisse) wird ein hoher Grad an <i>statistischer Validität</i> angenommen, wenn die Reliabilität und <a href="Trennsch%C3%A4rfe_eines_Tests" title="Trennschärfe eines Tests">Teststärke</a> der Messinstrumente und gewählten <a href="Statistik" title="Statistik">statistischen Verfahren</a> hoch ist und allgemein die <a href="Klassische_Testtheorie" title="Klassische Testtheorie">Fehlervarianz</a> begrenzt wurde, die mathematischen Annahmen der statistischen Methoden nicht verletzt wurden und nicht einzelne Signifikanzen (zum Beispiel aus einer <a href="Korrelationsmatrix" title="Korrelationsmatrix">Korrelationsmatrix</a>) „herausgefischt“ wurden (<i>Fishing</i>).
</p>
<div class="mw-heading mw-heading3"><h3 id="Interne_Validität"><span id="Interne_Validit.C3.A4t"></span>Interne Validität</h3></div>
<p>Für Aussagen oder in empirischen Studien gezogene Schlussfolgerungen wird ein hoher Grad an <i>interner Validität</i> angenommen, wenn Alternativerklärungen für das Vorliegen oder die Höhe der gefundenen Effekte weitestgehend ausgeschlossen werden können. Interne Validität (oder <a href="Ceteris_paribus" title="Ceteris paribus">Ceteris-paribus</a>-Validität) liegt vor, wenn die Veränderung der <a href="Abh%C3%A4ngige_und_unabh%C3%A4ngige_Variable" title="Abhängige und unabhängige Variable">abhängigen Variable</a> eindeutig auf die Variation der unabhängigen Variable zurückgeführt werden kann (keine Alternativerklärung). Um dies zu gewährleisten, müssen Störvariablen kontrolliert bzw. durch verschiedene Methoden wie Elimination, Konstanthaltung und Parallelisierung ausgeschaltet werden. Damit die Effekte nicht auf Merkmale der <a href="Proband" title="Proband">Probanden</a> zurückgeführt werden können, müssen diese <a href="Randomisierung" title="Randomisierung">zufällig</a> den Versuchsbedingungen zugeteilt werden.
</p><p>Die interne Validität wird gefährdet durch:<sup id="cite_ref-Krauth_2000_6-1" class="reference"><a href="#cite_note-Krauth_2000-6"><span class="cite-bracket">[</span>6<span class="cite-bracket">]</span></a></sup>
</p>
<ul><li>Geschichte. Jedes ungeplante Ereignis zwischen zwei Messungen kann einen ungewollten Einfluss auf die Probanden haben. Beispiel: Bei der ersten Messung, vor der Behandlung mit einem neuen Antidepressivum, ist das Wetter kalt und regnerisch, bei der zweiten Messung, die eine Wirkung des Medikaments prüfen soll, ist das Wetter warm und sonnig.</li>
<li>Reifung. Probanden ändern sich allein durchs Älterwerden zwischen zwei Messungen.</li>
<li>Reaktivität. Probanden reagieren eventuell auf die Messungen selbst, zum Beispiel mit <a href="Habituation" title="Habituation">Habituation</a> oder <a href="Sensitivierung" title="Sensitivierung">Sensitivierung</a>, insbesondere wenn der Messvorgang unangenehm ist.</li>
<li>Veränderung beim Messinstrument. Während einer Studie können sich die Eigenschaften der Messinstrumente, einschließlich der messenden Personen, ändern. Diese können zum Beispiel durch Erfahrung genauer oder durch wachsende Langeweile ungenauer messen. Auch kann die abhängige Variable durch die Behandlung in einen Wertebereich gelangen, in dem das Messinstrument weniger genau ist. Dadurch kann es zu <a href="Boden-_und_Deckeneffekt" title="Boden- und Deckeneffekt">Boden- oder Deckeneffekten</a> kommen. Beispiel: Um die Wirkung eines kognitiven Trainings für Kinder zu messen, wird ein Intelligenztest verwendet. Das Training ist so erfolgreich, dass die Kinder bei der zweiten Messung alle die volle Punktzahl erreichen.</li>
<li><a href="Regression_zur_Mitte" title="Regression zur Mitte">Regression zur Mitte</a>. Dieses statistische <a href="Artefakt_(Diagnostik)" title="Artefakt (Diagnostik)">Artefakt</a> kann Behandlungseffekte überlagern, wenn man, zum Beispiel um Boden- oder Deckeneffekte zu verhindern, Probanden mit besonders hohen (oder niedrigen) Anfangswerten im betreffenden Merkmal von vornherein ausschließt.</li>
<li>Selektion durch mangelhafte Randomisierung. Ist die Zuordnung der Probanden zu den Versuchsbedingungen nicht zufällig, können sich Experimental- und <a href="Kontrollgruppe" title="Kontrollgruppe">Kontrollgruppe</a> schon vor der Behandlung unterscheiden, sodass die Messung des Behandlungseffektes verfälscht wird. Zudem können sich Geschichts-, Reifungs- und Instrumenteneffekte auf die Gruppen in unterschiedlicher Weise auswirken.</li>
<li>Ausfall. Wenn Probanden während der Studie wegfallen, kann dies an der Behandlung liegen. Die bei der zweiten Messung kleineren Gruppen sind Ergebnis einer ungewollten Selektion.</li>
<li>Richtung des Kausalschlusses. Ein Kausalzusammenhang zwischen unabhängiger und abhängiger Variable wird zweifelhaft, wenn (in einer anderen Studie) ebenfalls ein Effekt von der abhängigen auf die unabhängige Variable gefunden wird und diese <a href="Korrelation" title="Korrelation">Korrelation</a> nicht durch eine dritte Variable erklärt werden kann.</li>
<li>Informationsaustausch. Wenn Probanden zwischen den Messungen interagieren (zum Beispiel „Ich glaube, ich gehöre zur Placebogruppe“), kann dies Auswirkungen auf den nächsten Messvorgang haben. Effekte der <a href="Konformit%C3%A4t" title="Konformität">Konformität</a> können die Effekte der Behandlung überlagern; oder eine Gruppe reagiert darauf, dass ihre Versuchsbedingungen viel unangenehmer sind als die der anderen Gruppe, zum Beispiel mit Kompensation oder Demotivation.</li>
<li><a href="Rosenthal-Effekt" title="Rosenthal-Effekt">Rosenthal-Effekte</a>. Der Versuchsleiter verrät unbewusst durch Gestik, Mimik und Wortwahl mehr über das Experiment, als die Versuchsperson wissen darf. Dabei lassen sich <a href="Autosuggestion" title="Autosuggestion">Autosuggestion</a> und <a href="Suggestion" title="Suggestion">Suggestion</a> unterscheiden. Bei ersterer erhebt der Versuchsleiter bei allem bewusstem Bemühen um Neutralität tendenziell Daten, die seine Vorerwartungen und Hypothesen stützen. Bei der Suggestion teilen sich diese Erwartungen der Versuchsperson mit, die gemäß den Vorerwartungen des Versuchsleiters handelt und passende Daten liefert (<i><span lang="en">good subject effect</span></i>).</li></ul>
<p>Im Englischen existiert hierzu die Eselsbrücke THIS MESS. Dieses <a href="Akronym" title="Akronym">Akronym</a> bezieht sich auf acht Faktoren, die Gefährdungen der internen Validität darstellen, nämlich <i>T</i>esting (vgl. Reaktivität), <i>H</i>istory (Geschichte), <i>I</i>nstrument change (Veränderung beim Messinstrument), <i>S</i>tatistical Regression toward the mean (Regression zur Mitte), <i>M</i>aturation (Reifung), <i>E</i>xperimental mortality (Ausfall), <i>S</i>election (Selektion durch mangelhafte Randomisierung) und <i>S</i>election Interaction (Wechselwirkung zwischen Selektion und einem anderen Faktor, z. B. Reifung nur in der Experimentalgruppe).<sup id="cite_ref-7" class="reference"><a href="#cite_note-7"><span class="cite-bracket">[</span>7<span class="cite-bracket">]</span></a></sup>
</p>
<div class="mw-heading mw-heading3"><h3 id="Externe_Validität"><span id="Externe_Validit.C3.A4t"></span>Externe Validität</h3></div>
<p>Die externe Validität – auch Allgemeingültigkeit, Verallgemeinerungsfähigkeit oder ökologische Validität (vgl. <a href="%C3%96kologischer_Fehlschluss" title="Ökologischer Fehlschluss">Ökologischer Fehlschluss</a>) – bezeichnet die Übereinstimmung von tatsächlichem und intendiertem Untersuchungsgegenstand. Grundidee ist hier die Frage nach der Generalisierbarkeit (Induktion). Nach der klassischen Sicht haben Aussagen oder in empirischen Studien gezogene Schlussfolgerungen einen hohen Grad an <i>externer Validität</i>, wenn sich (a) die Resultate auf die <a href="Grundgesamtheit" title="Grundgesamtheit">Grundgesamtheit</a> verallgemeinern lassen, für die die Studie konzipiert wurde, und (b) über das konkrete Setting der Studie hinaus auf andere Designs, Instrumente, Orte, Zeiten und Situationen übertragen lassen, also allgemeingültig, verallgemeinerungsfähig sind. Die häufigste Gefährdung der personenbezogenen externen Qualität (a) liegt in praktischen Problemen bei der Rekrutierung der Informationsträger, also der Personen, die befragt werden, oder der für ein <a href="Psychologisches_Experiment" title="Psychologisches Experiment">Experiment</a> benötigten <a href="Versuchsperson" class="mw-redirect" title="Versuchsperson">Versuchspersonen</a>. Ist ihre Teilnahme erzwungen oder freiwillig? Wie haben sie von der Teilnahmemöglichkeit erfahren (durch Zeitungsanzeige, Aushang usw.)? Was motiviert sie zur Teilnahme (interessiert sie das Thema, brauchen sie das Geld usw.)? Dies sind Filter, die die Qualität der Stichprobe einschränken können. Die häufigste Gefährdung der situationsbezogenen externen Qualität (b) liegt in der Künstlichkeit von Laborexperimenten.<sup id="cite_ref-8" class="reference"><a href="#cite_note-8"><span class="cite-bracket">[</span>8<span class="cite-bracket">]</span></a></sup>
</p><p>Die externe Validität erhöht sich mit jeder erfolgreichen Replikation der Befunde, denn durch die Wiederholung mit anderen Probanden (Altersgruppe, Geschlecht, Kultur usw.) oder Variationen der Versuchsbedingungen werden die Einschränkungen für die Gültigkeit der Befunde geringer. Beispiel: Solange <a href="Iwan_Petrowitsch_Pawlow" title="Iwan Petrowitsch Pawlow">Pawlow</a> nur gezeigt hatte, dass Hunden beim Erklingen einer Glocke das Wasser im Munde zusammenläuft, wenn die Glocke zuvor oft genug gleichzeitig mit der Gabe von Futter erklang, hat er eben nur das gezeigt. Vom Phänomen der <a href="Klassische_Konditionierung" title="Klassische Konditionierung">klassischen Konditionierung</a> kann man erst sprechen, wenn viele Arten von Subjekten viele Arten von bedingten Reaktionen auf viele Arten von bedingten Reizen zeigen. Für die statistische Auswertung von Replikationsstudien steht die Methode der <a href="Metaanalyse" title="Metaanalyse">Metaanalyse</a> zur Verfügung.
</p><p>Aus dieser klassischen Sicht stehen interne und externe Validität im Widerstreit: Ein hohes Maß an interner Validität erreicht man am besten durch hochkontrollierte und deshalb recht künstliche (Labor-)Bedingungen. Besonders realitätsnahe <a href="Forschungsdesign" title="Forschungsdesign">Forschungsdesigns</a>, wie sie für eine möglichst hohe externe Validität ratsam scheinen, bergen hingegen die Gefahr unkontrollierbarer oder übersehener Störeinflüsse. Aus einer <a href="Deduktion" title="Deduktion">deduktivistischen</a> Perspektive ist dies jedoch nur ein scheinbarer Widerspruch. Da beide Kriterien aus einer <a href="Induktivismus" title="Induktivismus">induktivistischen Forschungslogik</a> heraus entwickelt wurden, steht die Generalisierung empirischer Befunde (bspw. aus einem Experiment) im Vordergrund. Hier ist die Frage nach der Replizierbarkeit der Ergebnisse unter verschiedenen Bedingungen mit verschiedenen Stichproben eine sinnvolle Frage. Eine <a href="Kritischer_Rationalismus" title="Kritischer Rationalismus">deduktivistische Forschungslogik</a> verfolgt jedoch ein anderes Ziel. Hier wird versucht, eine (allgemeingültige) Theorie anhand einer speziellen Vorhersage zu <a href="Falsifikationismus" title="Falsifikationismus">falsifizieren</a>, nicht, wie in einer <a href="Logischer_Empirismus" title="Logischer Empirismus">empiristischen Forschungslogik</a>, eine Theorie durch genügend Beobachtungen zu verifizieren. Widerspricht nach dieser Logik die Beobachtung der Theorie, gilt diese als falsifiziert. Hierbei ist es irrelevant, ob die Ergebnisse in irgendeiner Weise „repräsentativ“ sind. Bestätigt sich die Vorhersage einer Theorie in einem Experiment, gilt die Theorie als bewährt, muss aber weiteren Prüfungen unterzogen werden. Einwände, die die Gültigkeit der Ergebnisse des Experiments in Frage stellen, sind Einwände gegen die interne Validität des Experiments.
</p><p>Das Forschungsdesign hat einen großen Einfluss auf die Zulässigkeit und Gültigkeit der Kausalschlüsse, darum werden die Validitäten bei <a href="Experiment" title="Experiment">experimentellen</a> und <a href="Quasi-Experiment" title="Quasi-Experiment">quasi-experimentellen</a> Forschungsdesigns immer kritisch hinterfragt.
</p>
<div class="mw-heading mw-heading2"><h2 id="Validität_in_der_biologischen_Nomenklatur"><span id="Validit.C3.A4t_in_der_biologischen_Nomenklatur"></span>Validität in der biologischen Nomenklatur</h2></div>
<p>Der Begriff „Validität“ bezieht sich in der <a href="Nomenklatur_(Biologie)" title="Nomenklatur (Biologie)">biologischen Nomenklatur</a> auf die formale Gültigkeit eines <a href="Taxon" title="Taxon">Taxons</a> (eine systematische Einheit von Lebewesen). Gültigkeit erlangt ein Taxon wenn beispielsweise deren <a href="Erstbeschreibung" title="Erstbeschreibung">Erstbeschreibung</a> den entsprechenden formalen Ansprüchen genügt (in der Botanik als „<a href="G%C3%BCltige_Publikation" title="Gültige Publikation">gültige Publikation</a>“ bezeichnet). Diese formalen Ansprüche sind in den einzelnen Bereichen der biologischen Nomenklatur erfüllt, wenn die jeweiligen Regel eingehalten worden sind. In der botanischen Nomenklatur sind diese im <a href="Internationaler_Code_der_Nomenklatur_f%C3%BCr_Algen%2C_Pilze_und_Pflanzen" title="Internationaler Code der Nomenklatur für Algen, Pilze und Pflanzen">Internationalen Code der Nomenklatur für Algen, Pilze und Pflanzen</a> (ICNafp) geregelt,<sup id="cite_ref-9" class="reference"><a href="#cite_note-9"><span class="cite-bracket">[</span>9<span class="cite-bracket">]</span></a></sup> in der zoologischen Nomenklatur in den <a href="Internationale_Regeln_f%C3%BCr_die_Zoologische_Nomenklatur" title="Internationale Regeln für die Zoologische Nomenklatur">Internationalen Regeln für die Zoologische Nomenklatur</a> (ICZN). Für weitere Regelwerke siehe auch <a href="Nomenklatur_(Biologie)#Internationale_Regelwerke_zur_Nomenklatur" title="Nomenklatur (Biologie)">Internationale Regelwerke zur Nomenklatur</a>. Diese Regeln werden von entsprechenden Kommissionen aufgestellt und weiterentwickelt. Im Falle der zoologische Nomenklatur ist dies die <a href="International_Commission_on_Zoological_Nomenclature" title="International Commission on Zoological Nomenclature">International Commission on Zoological Nomenclature</a>.
Valide (gültige) Taxa können außer durch Erstbeschreibungen auch durch Wiedererlangung der Gültigkeit von irrtümlich <a href="Synonym_(Taxonomie)" title="Synonym (Taxonomie)">synonymisierten</a> Taxa entstehen. In diesen Fällen wird dies als Revalidisierung bezeichnet. Auch Neukombinationen von mindestens <a href="Bin%C3%A4re_Nomenklatur" class="mw-redirect" title="Binäre Nomenklatur">binären Namen</a> können zu validen Taxa führen, z. B. durch die Einordnung einer <a href="Art_(Biologie)" title="Art (Biologie)">Art</a> in eine andere <a href="Gattung_(Biologie)" title="Gattung (Biologie)">Gattung</a>. Außerdem können durch Änderung der <a href="Rangstufe_(Zoologie)" class="mw-redirect" title="Rangstufe (Zoologie)">Rangstufe</a> neue Taxa entstehen. So kann beispielsweise eine <a href="Unterfamilie" class="mw-redirect" title="Unterfamilie">Unterfamilie</a> in den Rang einer <a href="Familie_(Biologie)" title="Familie (Biologie)">Familie</a> erhoben werden. Umgekehrt kann die Validität eines Taxons verloren gehen, etwa wenn es als Synonym zu einem Taxon erkannt wird, welches nach den gültigen Regeln Priorität hat. Auch durch die Veränderung einer Rangstufe kann die Validität verloren gehen. Aufgrund formaler Mängel bei der Erstbeschreibung eines Taxons kann dieses von der jeweils zuständigen Kommission als nicht valide eingestuft werden. Derartige Namen werden als <a href="Nomen_nudum" title="Nomen nudum">Nomen nudum</a> bezeichnet. Jede vom <a href="Autor_(Zoologie)" title="Autor (Zoologie)">Autor</a> beabsichtigte Änderung des Status eines Taxons muss seit 1999 in der entsprechenden Veröffentlichung gekennzeichnet werden, etwa als "<a href="Spec." class="mw-redirect" title="Spec.">spec.</a> nov." (species nova) oder "n. sp." für neue Art, "stat. rev." (status revidiert) oder "rev. stat." für wiederhergestellte, somit wieder valide Taxa, als "comb. nov." oder "n. comb." für neukombinierte, mindestens binominale Taxa. Aber auch für Taxa, die ihre Gültigkeit verloren haben, muss dies gekennzeichnet werden, beispielsweise als "n. syn." oder "syn. nov." für neues Synonym. In welcher Art die Kennzeichnung genau erfolgen soll, ist nicht genau definiert, allerdings muss sie eindeutig und gebräuchlich sein.<sup id="cite_ref-10" class="reference"><a href="#cite_note-10"><span class="cite-bracket">[</span>10<span class="cite-bracket">]</span></a></sup>
</p>
<div class="mw-heading mw-heading2"><h2 id="Literatur">Literatur</h2></div>
<ul><li><a href="Donald_T._Campbell" title="Donald T. Campbell">D. T. Campbell</a>, D. W. Fiske: <i>Convergent and discriminant validation by the multitrait-multimethod matrix.</i> In: <i><a href="Psychological_Bulletin" title="Psychological Bulletin">Psychological Bulletin</a>.</i> 56, 1959, S. 81–105.</li>
<li><a href="Andreas_Diekmann" title="Andreas Diekmann">Andreas Diekmann</a>: <i>Empirische Sozialforschung.</i> 18. Auflage, Reinbek bei Hamburg 2007.</li>
<li>R. M. Liebert, L. L. Liebert: <i>Science and behavior. An introduction to methods of psychological research.</i> Prentice Hall, Englewood Cliffs, NJ 1995.</li>
<li><a href="Rainer_Schnell" title="Rainer Schnell">Rainer Schnell</a>, <a href="Paul_B._Hill" title="Paul B. Hill">Paul B. Hill</a>, Elke Esser: <i>Methoden der Empirischen Sozialforschung.</i> 8., unveränderte Auflage, Oldenbourg Verlag, München 2008.</li>
<li>W. Shadish, T. Cook, D. Campbell: <i>Experimental and Quasi-Experimental Designs for Generalized Causal Inference.</i> Houghton Mifflin, Boston 2002.</li></ul>
<div class="mw-heading mw-heading2"><h2 id="Weblinks">Weblinks</h2></div>
<div class="sisterproject" style="margin:0.1em 0 0 0;"><span class="noviewer" style="display:inline-block; line-height:10px; min-width:1.6em; text-align:center;" aria-hidden="true" role="presentation"><span class="mw-default-size" typeof="mw:File"><span title="Wiktionary"></span></span></span><b><a href="https://de.wiktionary.org/wiki/Validit%C3%A4t" class="extiw external" title="wikt:Validität">Wiktionary: Validität</a></b> – Bedeutungserklärungen, Wortherkunft, Synonyme, Übersetzungen</div>
<div class="mw-heading mw-heading2"><h2 id="Einzelnachweise">Einzelnachweise</h2></div>
<ol class="references">
<li id="cite_note-1"><span class="mw-cite-backlink"><a href="#cite_ref-1">↑</a></span> <span class="reference-text">Lienert und Raatz 1994 nach <a rel="nofollow" class="external text" href="https://portal.hogrefe.com/dorsch/validitaet-1/">Validität im DORSCH Lexikon für Psychologie</a>.</span>
</li>
<li id="cite_note-2"><span class="mw-cite-backlink"><a href="#cite_ref-2">↑</a></span> <span class="reference-text">Fisseni, Hermann-Josef: Lehrbuch der psychologischen Diagnostik, 3. Auflage, Göttingen u. a. 2004, S. 62 f.</span>
</li>
<li id="cite_note-3"><span class="mw-cite-backlink"><a href="#cite_ref-3">↑</a></span> <span class="reference-text">Fisseni, Hermann-Josef: Lehrbuch der psychologischen Diagnostik, 3. Auflage, Göttingen u. a. 2004, S. 62 f. und Brockhaus Psychologie, 2. Auflage, Mannheim 2009.</span>
</li>
<li id="cite_note-4"><span class="mw-cite-backlink"><a href="#cite_ref-4">↑</a></span> <span class="reference-text">G. A. Lienert, U. Raatz: <i>Testaufbau und Testanalyse.</i> 5., völlig neubearbeitete und erweiterte Auflage, Beltz, Weinheim 1994, S. 220.</span>
</li>
<li id="cite_note-5"><span class="mw-cite-backlink"><a href="#cite_ref-5">↑</a></span> <span class="reference-text"><a href="Gustav_A._Lienert" title="Gustav A. Lienert">Gustav A. Lienert</a>: <i>Testaufbau und Testanalyse.</i> Psychologie Verlags Union, 4. Auflage, 1989, S. 256.</span>
</li>
<li id="cite_note-Krauth_2000-6"><span class="mw-cite-backlink">↑ <sup><a href="#cite_ref-Krauth_2000_6-0">a</a></sup> <sup><a href="#cite_ref-Krauth_2000_6-1">b</a></sup></span> <span class="reference-text">Joachim Krauth: <i>Experimental Design</i>. Elsevier/Saunders 2000. ISBN 0-444-50637-3.</span>
</li>
<li id="cite_note-7"><span class="mw-cite-backlink"><a href="#cite_ref-7">↑</a></span> <span class="reference-text">P. M. Wortman: <cite style="font-style:italic">Evaluation research – A methodological perspective</cite>. In: <cite style="font-style:italic">Annual Review of Psychology</cite>. 34. Jahrgang, 1983, <span style="white-space:nowrap">S.<span style="display:inline-block;width:.2em"> </span>223–260</span>, <a href="Digital_Object_Identifier" title="Digital Object Identifier">doi</a>:<span class="uri-handle" style="white-space:nowrap"><a rel="nofollow" class="external text" href="https://doi.org/10.1146/annurev.ps.34.020183.001255">10.1146/annurev.ps.34.020183.001255</a></span>.<span class="Z3988" title="ctx_ver=Z39.88-2004&rft_val_fmt=info%3Aofi%2Ffmt%3Akev%3Amtx%3Abook&rfr_id=info:sid/de.wikipedia.org:Validit%C3%A4t&rft.atitle=Evaluation+research+-+A+methodological+perspective&rft.au=P.+M.+Wortman&rft.btitle=Annual+Review+of+Psychology&rft.date=1983&rft.doi=10.1146%2Fannurev.ps.34.020183.001255&rft.genre=book&rft.pages=223-260&rft.volume=34.+Jahrgang" style="display:none"> </span></span>
</li>
<li id="cite_note-8"><span class="mw-cite-backlink"><a href="#cite_ref-8">↑</a></span> <span class="reference-text"><a href="Elliot_Aronson" title="Elliot Aronson">E. Aronson</a>, T. D. Wilson, R. M. Akert: <i>Sozialpsychologie</i>. Pearson Studium, 6. Auflage 2008, ISBN 978-3-8273-7359-5, S. 42 f.</span>
</li>
<li id="cite_note-9"><span class="mw-cite-backlink"><a href="#cite_ref-9">↑</a></span> <span class="reference-text">Paul van Rijckevorsel: <a rel="nofollow" class="external text" href="https://www.iapt-taxon.org/historic/index.htm"><i>Overview of editions of the Code.</i></a> International Association for Plant Taxonomy. November 2018, abgerufen am 2. Januar 2021.</span>
</li>
<li id="cite_note-10"><span class="mw-cite-backlink"><a href="#cite_ref-10">↑</a></span> <span class="reference-text">Otto Kraus: <i>Internationale Regeln für die Zoologische Nomenklatur</i>, Goecke & Evers, Keltern-Weiler, 4. Auflage, 2000, ISBN 3-931374-36-X</span>
</li>
</ol>
<div class="hintergrundfarbe1 rahmenfarbe1 navigation-not-searchable normdaten-typ-s" style="border-style: solid; border-width: 1px; clear: left; margin-bottom:1em; margin-top:1em; padding: 0.25em; overflow: hidden; word-break: break-word; word-wrap: break-word;" id="normdaten">
<div style="display: table-cell; vertical-align: middle; width: 100%;">
<div>
Normdaten (Sachbegriff): <a href="Gemeinsame_Normdatei" title="Gemeinsame Normdatei">GND</a>: <span class="-print"><a rel="nofollow" class="external text" href="https://d-nb.info/gnd/4062305-1">4062305-1</a></span> </div>
</div></div></div><!--htdig_noindex--><div><div class="zim-footer">
Dieser Artikel wurde von <a class="external text" title="Zuletzt bearbeitet am 2025-03-06" href="https://de.wikipedia.org/wiki/?title=Validit%C3%A4t&oldid=253958781">Wikipedia</a> herausgegeben. Der Text ist unter <a class="external text" href="https://creativecommons.org/licenses/by-sa/4.0/deed.de">Creative Commons Attribution-Share Alike 4.0</a> verfügbar, sofern nicht anders angegeben. Für die Mediendateien können zusätzliche Bedingungen gelten.
</div>
</div><!--/htdig_noindex--></div>
</div>
</main>
</div>
</div>
</div>
<script src="./_webp_/webpHandler.js"></script>
</body></html>